你买了一台 AI 迷你主机,或者正在考虑买,但心里有个疑问一直没搞明白:这东西能不能在完全断网的环境下用?如果办公室断网了、出差没 Wi-Fi、或者我单位根本就不能连外网——AI 还能用吗?
这是很多企业 IT 采购和个人用户最关心的问题之一。答案是明确的:AI 迷你主机可以完全离线运行大模型,无需任何网络连接。
AI 迷你主机从设计上就支持离线运行,不依赖外网。
原因很简单:AI 迷你主机的算力在本地(NPU/GPU/核显),模型存在本地硬盘,推理框架也在本地运行。没有任何一个环节需要联网。
| 环节 | 是否依赖网络 | 说明 |
|---|---|---|
| 加载模型到内存 | 不需要 | 模型在本地 SSD/eMMC,直接读取 |
| AI 推理计算 | 不需要 | NPU/GPU 本地计算 |
| 对话交互 | 不需要 | 本地输入输出 |
| 模型激活验证 | 不需要 | 开源模型无需在线激活 |
| 系统启动 | 不需要 | 无需联网验证 |
唯一的例外是首次部署:如果设备出厂没有预装模型,首次下载需要联网。但一旦模型下载到本地,后续完全离线可用。
AI 推理需要的是“算力”,不是“网络”。
x86 系列(PB1001/PB1202):靠核显(GPU)算力推理
x86+NPU 系列(PB1301/PB1501):靠 NPU 算力推理
ARM+NPU 系列(PB0601/PB0801):靠 NPU 算力推理
这些算力芯片焊在主板上,不需要连接任何云端服务器。
大模型本质上是一个文件(如 Qwen2.5-7B-Q4 约 4.5GB),存放在设备的 SSD 或 eMMC 中。推理时,模型被加载到内存中运行,所有计算在设备内部完成——不会“上传”任何数据,不需要“联网搜索”。
Ollama、LM Studio、RKNN 等推理框架都是本地软件,安装后完全离线可用,不需要连接任何云端 API。
| 对比维度 | 联网使用 | 离线使用 |
|---|---|---|
| 模型加载 | 相同 | 相同 |
| 推理速度 | 相同(硬件决定) | 相同(硬件决定) |
| 生成质量 | 相同 | 相同 |
| 数据隐私 | 数据在本地 | 数据在本地 |
| 首次下载模型 | 需要 | 无法下载 |
| 后续使用 | 正常 | 完全正常 |
关键结论:联网仅影响“首次下载模型”,不影响“运行模型”。一旦模型下载完成,离线状态下的体验与联网状态完全一致。
| 型号 | 架构 | 算力来源 | 离线运行 | 出厂预装模型 | 推荐场景 |
|---|---|---|---|---|---|
| PB1001 | x86 | Vega 8 核显 | 支持 | 可选预装 | 入门离线 AI 办公 |
| PB1202 | x86 | Radeon 660M | 支持 | 可选预装 | 离线 7B 模型推理 |
| PB1301 | x86 | 50 TOPS NPU | 支持 | 可选预装 | 离线 NPU 加速推理 |
| PB1401 | x86 | RTX 3060 | 支持 | 可选预装 | 离线 CUDA AI 开发 |
| PB1501 | x86 | 50 TOPS + 128GB | 支持 | 可选预装 | 离线 70B 大模型 |
| PB0601 | ARM | 6 TOPS NPU | 支持 | 可选预装 | 政企无外网批量部署 |
| PB0801 | ARM | 6 TOPS NPU(三核) | 支持 | 可选预装 | 政企无外网复杂任务 |
如果你已经有一台 AI 迷你主机,想验证它是否真的支持离线运行,按以下步骤操作:
第一步:通电开机
不插网线,不通 Wi-Fi
设备正常启动进入桌面
第二步:打开推理软件
打开 Ollama 或 LM Studio
软件正常启动,无联网报错
第三步:加载本地模型
选择已下载的模型(如 Qwen2.5-7B)
模型正常加载到内存
第四步:发送对话
输入问题,模型正常回复
推理速度与联网时相同
全部通过 = 完全离线可用
如果设备出厂预装了模型(PB0601/PB0801 默认预装,其他型号可选),上述步骤可以直接跑通。如果设备没有预装模型,需要先联网下载一次(下载完成后即可永久离线使用)。
政企单位对“离线 AI”的需求最为刚性——数据不能出内网,设备不能连外网,AI 还要照常工作。
| 场景 | 需求 | 解决方案 |
|---|---|---|
| 政务公文起草 | 数据不出政务内网 | 部署 PB0601,预装 Qwen2.5-7B |
| 国企内部知识库 | 规章制度不上云 | 部署 PB0801,本地 RAG |
| 军工文档分析 | 物理隔离网络 | PB0801,物理断网运行 |
| 金融合规审查 | 客户数据本地处理 | PB1301/PB1501,x86+NPU 离线 |
单机部署:每台设备分配给一个用户,本地使用
text
[用户] → [AI 迷你主机] → [本地推理] ↑ 所有数据在本地
内网共享部署:一台设备部署在内网,供多人调用
text
[员工A] → [内网交换机] [员工B] → [内网交换机] → [AI 迷你主机] → [本地推理] [员工C] → [内网交换机] ↑ 所有数据在内网
两种方式均无需外网,部署完成后可物理断开外网。
A:不需要。 AI 迷你主机不依赖云端激活,通电即可使用。如果预装了模型,完全不联网也能直接运行。如果需要自己下载模型,首次下载需联网,下载完成后永久离线可用。
A:不会。 推理速度由 NPU/GPU 算力决定,与网络无关。离线状态下的 tokens/秒 与联网状态完全一致。
A:可以。技术团队可通过 U 盘或内网文件服务器导入新模型。华一精品也提供后续模型更新服务(通过内网离线包方式交付)。
A:
单机部署 / 批量走量:PB0601(¥1,750) ,6 TOPS NPU,10W 功耗,预装系统+模型
多任务并发 / 复杂模型:PB0801(¥1,950) ,三核 NPU 并行
需要 Windows + x86 生态:PB1301 或 PB1501
A:
本地 7B/13B 模型:能力相当于 GPT-3.5 到 GPT-4 早期水平,可满足公文起草、知识库问答、文档摘要等绝大多数企业任务
数据安全:本地部署 > 云端 API(数据不出本地)
长期成本:本地部署 ≈ 一次性投入,云端 API = 持续月费
对于不追求“地表最强 AI”的企业日常办公场景,本地 7B/13B 模型的能力已经足够。